Micron Document
<!DOCTYPE html>
<html class="client-nojs vector-feature-language-in-header-enabled vector-feature-language-in-main-page-header-disabled vector-feature-page-tools-pinned-disabled vector-feature-toc-pinned-clientpref-0 vector-toc-not-available vector-feature-main-menu-pinned-disabled vector-feature-limited-width-clientpref-1 vector-feature-limited-width-content-enabled vector-feature-custom-font-size-clientpref-1 vector-feature-appearance-pinned-clientpref-0 vector-feature-night-mode-enabled skin-theme-clientpref-os vector-sticky-header-enabled" lang="fr" dir="ltr"><head>
<meta charset="UTF-8">
<title>Web profond</title>
<meta name="viewport" content="width=device-width, initial-scale=1.0">
<link rel="icon" type="image/png" href="./_res_/favicon.png">
<link rel="canonical" href="https://fr.wikipedia.org/wiki/Web_profond"> <link href="./_mw_/ext.cite.styles.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.wikimediamessages.styles.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.icons.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.search.codex.styles.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.styles.css" rel="stylesheet" type="text/css">
<meta name="ResourceLoaderDynamicStyles" content="">
<link rel="stylesheet" type="text/css" href="./_mw_/site.styles.css">
<link rel="stylesheet" type="text/css" href="./_mw_/noscript.css">
<link rel="stylesheet" type="text/css" href="./_res_/footer.css">
<link rel="stylesheet" type="text/css" href="./_res_/vector-2022.css">
</head>
<body class="skin--responsive skin-vector skin-vector-search-vue mediawiki ltr sitedir-ltr mw-hide-empty-elt ns-0 ns-subject page-Web_profond rootpage-Web_profond skin-vector-2022 action-view">
<div class="mw-page-container">
<div class="mw-page-container-inner">
<div class="mw-content-container">
<main id="content" class="mw-body">
<header class="mw-body-header vector-page-titlebar">
<h1 id="firstHeading" class="firstHeading mw-first-heading"><span class="mw-page-title-main">Web profond</span></h1>
</header>
<a id="top"></a>
<div id="bodyContent" class="vector-body ve-init-mw-desktopArticleTarget-targetContainer" aria-labelledby="firstHeading" data-mw-ve-target-container="">
<div id="contentSub">
<div id="mw-content-subtitle"></div>
</div>
<div id="mw-content-text" class="mw-body-content mw-content-ltr" lang="fr" dir="ltr"><div class="mw-content-ltr mw-parser-output" lang="fr" dir="ltr">
<p>Le <b>web profond</b><sup id="cite_ref-GDT_1-0" class="reference"><a href="#cite_note-GDT-1"><span class="cite-bracket">[</span>1<span class="cite-bracket">]</span></a></sup> (<i><span class="lang-en" lang="en">deep web</span></i> en anglais), aussi appelé <b>toile profonde</b><sup id="cite_ref-JORF_2-0" class="reference"><a href="#cite_note-JORF-2"><span class="cite-bracket">[</span>2<span class="cite-bracket">]</span></a></sup> ou <b>web invisible</b><sup id="cite_ref-GDT_1-1" class="reference"><a href="#cite_note-GDT-1"><span class="cite-bracket">[</span>1<span class="cite-bracket">]</span></a></sup> au Québec <sup id="cite_ref-jep/07-01_3-0" class="reference"><a href="#cite_note-jep/07-01-3"><span class="cite-bracket">[</span>3<span class="cite-bracket">]</span></a></sup>, est l’ensemble des contenus accessibles sur <a href="World_Wide_Web" title="World Wide Web">Internet</a> mais non indexés par les <a href="Liste_de_moteurs_de_recherche#Moteurs_de_recherche_Web" title="Liste de moteurs de recherche">principaux moteurs de recherche généralistes</a><sup id="cite_ref-4" class="reference"><a href="#cite_note-4"><span class="cite-bracket">[</span>4<span class="cite-bracket">]</span></a></sup>.
Contrairement au <a href="Web_surfacique" title="Web surfacique">web de surface</a>, qui regroupe les <a href="Page_web" title="Page web">pages visibles</a> via une recherche classique, le <b>web profond</b> comprend toutes celles nécessitant une authentification, un accès restreint ou générées dynamiquement à la demande. Il englobe notamment des bases de données académiques, gouvernementales et scientifiques, ainsi que des plateformes bancaires, des réseaux internes d’entreprises et des services en ligne protégés par identifiant et mot de passe (boîte mail, cloud, <a href="Streaming" title="Streaming">streaming</a>, etc.).
</p><p>Dans l'<a href="World_Wide_Web#Architecture" title="World Wide Web">architecture du web</a>, le web profond est ainsi la partie sous-jacente essentielle au bon fonctionnement du web de surface, garantissant entre autres la confidentialité et la sécurité des informations en ligne.
</p><p>Il arrive fréquemment que le terme soit employé de manière inappropriée pour désigner les contenus difficilement accessibles, susceptibles d'être choquants, voire illégaux, présents sur le <a href="Dark_web" title="Dark web">dark web</a>, alors que ce dernier n'est qu'une infime partie du web profond.
</p>

<div class="mw-heading mw-heading2"><h2 id="Définition"><span id="D.C3.A9finition"></span>Définition</h2></div>
<p>En <a href="2001" title="2001">2001</a>, Michael K. Bergman compose l'expression <i>deep web</i> pour le vocabulaire des <a href="Moteur_de_recherche" title="Moteur de recherche">moteurs de recherche</a><sup id="cite_ref-wright2009_5-0" class="reference"><a href="#cite_note-wright2009-5"><span class="cite-bracket">[</span>5<span class="cite-bracket">]</span></a></sup>. Ce terme est construit par opposition au <a href="Web_surfacique" title="Web surfacique">web surfacique</a> ou <i>web référencé</i>. Il représente la partie de la toile qui n'est pas référencée par les <a href="Liste_de_moteurs_de_recherche#Moteurs_de_recherche_Web" title="Liste de moteurs de recherche">moteurs de recherche généralistes</a> (certains moteurs, tels que <a href="BASE_(moteur_de_recherche)" title="BASE (moteur de recherche)">BASE</a>, prennent en compte cette partie du réseau). Le <i>deep web</i> se rapporte à une dimension technique indépendamment du contenu.
</p><p>Tous les sites web peuvent contenir des pages dans la <i>toile profonde</i>. On y trouve notamment les <a href="Messagerie_web" title="Messagerie web">messagerie web</a>, les banques en ligne, ou des sites à accès restreint, voire partiellement ou intégralement payant (voir <a href="#Raisons_de_la_non-indexation">Raisons de la non-indexation</a>). Il y a aussi les pages qui changent en fonction de l'utilisateur, comme les réseaux sociaux.
</p><p>«&nbsp;Il convient de distinguer la toile profonde (deep web) de l'internet clandestin.&nbsp;»<sup id="cite_ref-6" class="reference"><a href="#cite_note-6"><span class="cite-bracket">[</span>6<span class="cite-bracket">]</span></a></sup> (en anglais darknet), un <a href="R%C3%A9seau_superpos%C3%A9" title="Réseau superposé">réseau superposé</a> avec des fonctions d'anonymisation. La toile profonde est un contenu indexable mais non indexé de la toile, comme la page d'un compte bancaire. Elle n'est pas non plus un <a href="Anonymat_sur_Internet#Anonymisation_par_chaînage_de_serveur_mandataire_(proxy)" title="Anonymat sur Internet">réseau d'anonymisation</a> (les <a href="Service_web" title="Service web">services web</a> auxquels on peut accéder via des outils tels <a href="Tor_(r%C3%A9seau)" title="Tor (réseau)">Tor</a>, <span class="lang-en" lang="en"><a href="Freenet" class="mw-redirect" title="Freenet">Freenet</a></span>, <a href="I2P" title="I2P">I2P</a>…).
</p>

<div class="mw-heading mw-heading2"><h2 id="Confusion_dans_l'utilisation_du_mot_deep_web"><span id="Confusion_dans_l.27utilisation_du_mot_deep_web"></span>Confusion dans l'utilisation du mot deep web</h2></div>
<p>L'expression «&nbsp;<i><span class="lang-en" lang="en">deep web</span></i>&nbsp;» est régulièrement utilisée dans les médias pour parler de sites web dont le contenu ou les services seraient choquants ou illégaux<sup id="cite_ref-7" class="reference"><a href="#cite_note-7"><span class="cite-bracket">[</span>7<span class="cite-bracket">]</span></a></sup><sup class="reference cite_virgule">,</sup><sup id="cite_ref-8" class="reference"><a href="#cite_note-8"><span class="cite-bracket">[</span>8<span class="cite-bracket">]</span></a></sup><sup class="reference cite_virgule">,</sup><sup id="cite_ref-9" class="reference"><a href="#cite_note-9"><span class="cite-bracket">[</span>9<span class="cite-bracket">]</span></a></sup>. Les médias ne parlent alors plus seulement de sites cachés ou invisibles au sens technique du référencement par les moteurs de recherche mais dans un sens plus social pour évoquer leur faible visibilité.
</p><p>La confusion est régulière y compris dans la presse généraliste comme en <time class="nowrap" datetime="2017-07" data-sort-value="2017-07">juillet 2017</time> lorsque certains journaux <sup id="cite_ref-10" class="reference"><a href="#cite_note-10"><span class="cite-bracket">[</span>10<span class="cite-bracket">]</span></a></sup><sup class="reference cite_virgule">,</sup><sup id="cite_ref-11" class="reference"><a href="#cite_note-11"><span class="cite-bracket">[</span>11<span class="cite-bracket">]</span></a></sup> reprennent une information de l'<a href="Agence_France-Presse" title="Agence France-Presse">Agence France-Presse</a> et définissent de manière erronée le <i>deep web</i> comme étant «&nbsp;seulement accessible au moyen de réseaux spécifiques».
</p><p>La confusion avec le <a href="Dark_web" title="Dark web">dark web</a> est parfois complète comme dans un article publié en <time class="nowrap" datetime="2017-03" data-sort-value="2017-03">mars 2017</time> sur rtl.be où l'on peut lire que «&nbsp;le <i>deep web</i> se trouve [...] sur un autre réseau, parallèle à internet. Les adresses URL des sites se terminent par .onion [...]&nbsp;»<sup id="cite_ref-12" class="reference"><a href="#cite_note-12"><span class="cite-bracket">[</span>12<span class="cite-bracket">]</span></a></sup> ce qui ne correspond qu'au <a href="Dark_web" title="Dark web">dark web</a> et plus précisément à <a href="Tor_(r%C3%A9seau)" title="Tor (réseau)">Tor</a>.
</p>
<div class="mw-heading mw-heading2"><h2 id="Ressources_profondes">Ressources profondes</h2></div>
<p>Les <a href="Robot_d'indexation" title="Robot d'indexation">robots d'indexation</a> sont des programmes utilisés par les moteurs de recherche pour parcourir le web. Afin de découvrir de nouvelles pages, ces robots suivent les <a href="Hyperlien" title="Hyperlien">hyperliens</a>. Les ressources profondes sont celles qui ne peuvent pas être atteintes facilement par les moteurs de recherche.
</p><p>Les ressources du web profond peuvent être classées dans une ou plusieurs des catégories suivantes&nbsp;:
</p>
<ul><li>contenu dynamique&nbsp;;</li>
<li>contenu non lié&nbsp;;</li>
<li>contenu à accès limité&nbsp;;</li>
<li>contenu de script&nbsp;;</li>
<li>format non indexable.</li></ul>
<p>(voir la section <i><a href="#Raisons_de_la_non-indexation">Raisons de la non-indexation</a></i> pour plus de précision).
</p>
<div class="mw-heading mw-heading2"><h2 id="Taille">Taille</h2></div>

<p>Une étude de juillet 2001 réalisée par l'entreprise <span class="lang-en" lang="en">BrightPlanet</span><sup id="cite_ref-jep/07-01_3-1" class="reference"><a href="#cite_note-jep/07-01-3"><span class="cite-bracket">[</span>3<span class="cite-bracket">]</span></a></sup> estimait que le web profond pouvait contenir 500&nbsp;fois plus de ressources que le web indexé par les moteurs de recherche. Ces ressources, en plus d'être volumineuses, notamment parce que la compression des fichiers y est moins importante, sont souvent de très bonne qualité.
</p><p>Il s'agit d'un ensemble de ressources connectées à Internet qui ne peuvent pas être trouvées par les moteurs de recherche, car elles ne sont pas indexées, par conséquent, le système DNS ne les trouvera pas. En d'autres termes, ce sont des machines qui n'ont pas de DNS associé, qui sont connectées à Internet mais qui ne peuvent pas être localisées et pour cela elles doivent utiliser des procédures spécifiques. Pour cette raison, les criminels se rendent sur le Web profond pour accéder à des forums pédophiles, par exemple.
</p><p>Les sites Web et les ressources ont une <a href="Adresse_IP" title="Adresse IP">adresse IP</a> spécifique et une chaîne de chiffres inintelligible que nous ne pourrons pas localiser parce qu'il s'agit de pages privées (ressources configurées pour ne pas apparaître publiquement) et parce qu'ils ont des caractéristiques techniques qui bloquent l'indexation (spiders ou crawlers qui sont des robots d'indexation).
</p><p>D'après le site spécialisé GinjFo, le <i>deep web</i> représenterait 96&nbsp;% de l'intégralité du web alors que le <i>web surfacique</i> ne représenterait que 4&nbsp;% du contenu<sup id="cite_ref-13" class="reference"><a href="#cite_note-13"><span class="cite-bracket">[</span>13<span class="cite-bracket">]</span></a></sup>.
</p><p>En <a href="2008" title="2008">2008</a>, le web invisible représenterait 70 à 75&nbsp;% de l'ensemble du <a href="Trafic_internet" class="mw-redirect" title="Trafic internet">trafic internet</a>, soit environ un <a href="Trilliard" title="Trilliard">trilliard</a> de <a href="Pages_web" class="mw-redirect" title="Pages web">pages web</a> non indexées<sup id="cite_ref-14" class="reference"><a href="#cite_note-14"><span class="cite-bracket">[</span>14<span class="cite-bracket">]</span></a></sup>.
</p>
<div class="mw-heading mw-heading2"><h2 id="Web_opaque">Web opaque</h2></div>
<p>Une partie très importante du web est théoriquement indexable, mais non indexée de fait par les moteurs. Certains auteurs<sup id="cite_ref-15" class="reference"><a href="#cite_note-15"><span class="cite-bracket">[</span>15<span class="cite-bracket">]</span></a></sup> parlent dans ce cas, pour le web non profond et non indexé, de <span class="citation">«&nbsp;web opaque&nbsp;»</span> (<i><span class="lang-en" lang="en">opaque web</span></i>) ou de <span class="citation">«&nbsp;web presque visible&nbsp;»</span> (<i><span class="lang-en" lang="en">nearly visible web</span></i>).
</p><p>Pour résumer, le web profond et le web opaque sont tous deux accessibles en ligne aux internautes et non indexés par les moteurs, mais le web opaque, lui, pourrait être indexé.
</p><p>Les <a href="Algorithme" title="Algorithme">algorithmes</a> des moteurs étant semblables (par exemple, <span class="lang-en" lang="en"><a href="PageRank" title="PageRank">PageRank</a></span>), les zones indexées se recoupent en partie d'un moteur de recherche à l'autre. Les ressources matérielles des robots d'indexation ne sont pas, malgré des moyens matériels importants, à même de suivre tous les liens théoriquement visibles par eux, que le web (gigantesque) contient.
</p><p>Une équipe de chercheurs allemands a étudié le comportement des robots d'indexation face à des sites contenant énormément de pages. Ils ont créé un site web composé de 2&nbsp;147&nbsp;483&nbsp;647&nbsp;pages (2<sup>31</sup> - 1). Ce site web étant un <a href="Arbre_binaire" title="Arbre binaire">arbre binaire</a>, il est très profond&nbsp;: il faut au minimum 31&nbsp;clics pour arriver à certaines pages. Ils ont laissé ce site en ligne, sans le modifier, pendant une année. Les résultats montrent que le nombre de pages indexées pour ce site, dans le meilleur des cas, ne dépasse pas 0,0049&nbsp;%.
</p><p>Afin de résoudre ce problème de volumétrie de pages à indexer pour un site donné, le moteur <a href="Google" title="Google">Google</a> a introduit en 2005 le <a href="Protocole_de_communication" title="Protocole de communication">protocole</a> <span class="lang-en" lang="en"><a href="Plan_de_site" title="Plan de site">sitemap</a></span>. Il permet, grâce à la mise à disposition du robot d'un fichier <span class="lang-en" lang="en">sitemap</span>, de gagner en efficacité pour l'indexation. Ce fichier est mis à la racine du site par l'administrateur du <a href="Site_web" title="Site web">site web</a>.
</p>
<div class="mw-heading mw-heading2"><h2 id="Raisons_de_la_non-indexation">Raisons de la non-indexation</h2></div>
<ul><li>Les sites contiennent de plus en plus de <a href="Page_web_dynamique" title="Page web dynamique">pages dynamiques</a>&nbsp;: les hyperliens de navigation sont générés à la demande et diffèrent d'une visite à l'autre.</li>
<li>Certains sites (ou partie de sites) ne sont pas liées par d'autres pages et ne peuvent donc pas être découvertes par les robots d'indexation (le seul moyen de les faire indexer est dès lors de demander explicitement cette indexation au moteur de recherche, ce qui est rarement fait, par ignorance de ce procédé). Ce contenu est connu comme des pages sans <i><span class="lang-en" lang="en">backlinks</span></i> (ou <i><span class="lang-en" lang="en">inlinks</span></i>).</li>
<li>Il faut parfois remplir convenablement un formulaire de critères de recherche pour pouvoir accéder à une page précise. C'est le cas de sites exploitant des banques de données.</li>
<li>Certains sites nécessitent une authentification (requérant un identifiant et un mot de passe) avant d'accéder au contenu réel&nbsp;: c'est le cas de sites payants et de sites avec des archives payantes (journaux en ligne, bases de données de météorologie,&nbsp;<abbr class="abbr" title="et cetera">etc.</abbr>).</li>
<li>Les pages Web peuvent, par leur conception, rendre difficile leur indexation. Elles peuvent en particulier contenir des <a href="%C3%89l%C3%A9ment_HTML" title="Élément HTML">éléments HTML</a> <tt><a href="%C3%89l%C3%A9ment_HTML#Jeu_de_cadres" title="Élément HTML">frameset</a></tt> au lieu des éléments classiques <tt><a href="%C3%89l%C3%A9ment_HTML#Éléments_racines" title="Élément HTML">body</a></tt>. Les balises consistant en un fichier robot.txt inséré dans le code d'une page permettent de protéger son <a href="Copyright" class="mw-redirect" title="Copyright">copyright</a>, de limiter les visites ou préserver le site d’accès trop fréquents. Or un robot n'est guère capable d'émettre des requêtes pertinentes&nbsp;; sa visite d'indexation se réduit donc aux seules pages accessibles en suivant des <a href="Uniform_Resource_Locator" title="Uniform Resource Locator">URL</a> statiques.</li>
<li>L'utilisation du langage <a href="JavaScript" title="JavaScript">JavaScript</a> (comme <a href="Ajax_(informatique)" title="Ajax (informatique)">Ajax</a>), mal compris, voire incompris par les robots<sup id="cite_ref-16" class="reference"><a href="#cite_note-16"><span class="cite-bracket">[</span>16<span class="cite-bracket">]</span></a></sup>, pour lier les pages entre elles constitue souvent un frein à leur indexation.</li>
<li>Le web invisible est également constitué des ressources utilisant des <a href="Format_de_donn%C3%A9es" title="Format de données">formats de données</a> incompréhensibles par les moteurs de recherche. Cela a été longtemps le cas du format <a href="Portable_Document_Format" title="Portable Document Format">PDF</a> ou ceux de <a href="Microsoft_Office" title="Microsoft Office">Microsoft Office</a> (Excel, Word, Power Point…), le seul format reconnu initialement étant le langage natif du Web, l’<a href="Hypertext_Markup_Language" title="Hypertext Markup Language">HTML</a>. Les grands moteurs de recherche (<a href="Google" title="Google">Google</a>, <a href="Yahoo!" title="Yahoo!">Yahoo!</a>, <a href="Bing_(moteur_de_recherche)" class="mw-redirect" title="Bing (moteur de recherche)">Bing</a>…) sont capables d'indexer avec plus ou moins d'efficacité les documents utilisant ces formats<sup id="cite_ref-17" class="reference"><a href="#cite_note-17"><span class="cite-bracket">[</span>17<span class="cite-bracket">]</span></a></sup><sup class="reference cite_virgule">,</sup><sup id="cite_ref-18" class="reference"><a href="#cite_note-18"><span class="cite-bracket">[</span>18<span class="cite-bracket">]</span></a></sup>. Google reconnaît les pages au format <a href="Adobe_Flash" title="Adobe Flash">flash</a><sup id="cite_ref-19" class="reference"><a href="#cite_note-19"><span class="cite-bracket">[</span>19<span class="cite-bracket">]</span></a></sup> depuis le début de 2008.</li>
<li>Les moteurs de recherche classiques n’indexent qu’entre 5 et 60&nbsp;% du contenu des sites accueillant de grandes bases de données&nbsp;: <a href="Internet_Movie_Database" title="Internet Movie Database">Internet Movie Database</a>, <a href="PubMed" title="PubMed">PubMed</a>, le <span class="lang-en" lang="en"><a href="National_Climatic_Data_Center" title="National Climatic Data Center">National Climatic Data Center</a></span> qui met en ligne une <a href="Base_de_donn%C3%A9es" title="Base de données">base de données</a> contenant 370&nbsp;000&nbsp;<abbr class="abbr" title="gibioctet">Gio</abbr>, alors que celle de la <a href="National_Aeronautics_and_Space_Administration" title="National Aeronautics and Space Administration">NASA</a> est de 220&nbsp;000&nbsp;<abbr class="abbr" title="gibioctet">Gio</abbr><sup id="cite_ref-20" class="reference"><a href="#cite_note-20"><span class="cite-bracket">[</span>20<span class="cite-bracket">]</span></a></sup>.</li>
<li>Les moteurs indexent partiellement les pages volumineuses&nbsp;: <a href="Google" title="Google">Google</a> et <a href="Yahoo!" title="Yahoo!">Yahoo!</a> se contentent de 500 kilooctets<sup id="cite_ref-21" class="reference"><a href="#cite_note-21"><span class="cite-bracket">[</span>21<span class="cite-bracket">]</span></a></sup>.</li></ul>
<div class="mw-heading mw-heading2"><h2 id="Web_privé"><span id="Web_priv.C3.A9"></span>Web privé</h2></div>
<p>Certaines pages sont inaccessibles aux robots du fait de la volonté de l'administrateur du site web. L'utilisation du fichier <a href="Protocole_d'exclusion_des_robots" title="Protocole d'exclusion des robots">robots.txt</a> notamment, mis à la racine d'un site web, permet de bloquer tout ou partie du site aux robots qui coopèrent, le site restant accessible aux internautes. Il est également possible d'utiliser l'<a href="%C3%89l%C3%A9ment_meta#L'attribut_robots" title="Élément meta">élément meta robot</a> dans le même but ainsi que pour empêcher de suivre des liens et interdire la mise en cache de pages (indépendamment de l'autorisation d'indexation). Ces pages sont alors parfois rangées dans une catégorie connexe à celle du web profond&nbsp;: le web privé (<i><span class="lang-en" lang="en">private web</span></i>).
</p>
<div class="mw-heading mw-heading2"><h2 id="Web_propriétaire"><span id="Web_propri.C3.A9taire"></span>Web propriétaire</h2></div>
<p><span class="need_ref" title="Ce passage nécessite une référence." style="cursor:help;">Le web propriétaire concerne les pages où il est nécessaire de s’identifier pour accéder au contenu. Le web propriétaire est compris dans le web profond.</span><sup class="need_ref_tag" style="padding-left:2px;">[réf.&nbsp;nécessaire]</sup>
</p>
<div class="mw-heading mw-heading2"><h2 id="Notes_et_références"><span id="Notes_et_r.C3.A9f.C3.A9rences"></span>Notes et références</h2></div>
<div class="references-small decimal" style=""><div class="mw-references-wrap mw-references-columns"><ol class="references">
<li id="cite_note-GDT-1"><span class="reference-text">Terme recommandé depuis 2019 au <a href="Qu%C3%A9bec" title="Québec">Québec</a>, cf. <span class="ouvrage">«&nbsp;<a rel="nofollow" class="external text" href="https://vitrinelinguistique.oqlf.gouv.qc.ca/redirection/ficheuid/8370264"><cite style="font-style:normal;">Web invisible</cite></a>&nbsp;», <i><a href="Grand_Dictionnaire_terminologique" title="Grand Dictionnaire terminologique">Grand Dictionnaire terminologique</a></i>, <a href="Office_qu%C3%A9b%C3%A9cois_de_la_langue_fran%C3%A7aise" title="Office québécois de la langue française">Office québécois de la langue française</a> <small style="line-height:1em;">(consulté le <time class="nowrap" datetime="2020-02-09" data-sort-value="2020-02-09">9 février 2020</time>)</small></span>.</span>
</li>
<li id="cite_note-JORF-2"><span class="mw-cite-backlink"><a href="#cite_ref-JORF_2-0">↑</a> </span><span class="reference-text">Terme recommandé depuis 2017 en <a href="France" title="France">France</a> par la Commission d’enrichissement de la langue française, cf. <span class="ouvrage">«&nbsp;<a rel="nofollow" class="external text" href="https://www.legifrance.gouv.fr/affichTexte.do?cidTexte=JORFTEXT000035638782&amp;dateTexte=&amp;categorieLien=id"><cite style="font-style:normal;">Vocabulaire de l'informatique et de l'internet (liste de termes, expressions et définitions adoptés) NOR: CTNR1725303K</cite></a>&nbsp;», sur <span class="italique"><a href="L%C3%A9gifrance" title="Légifrance">Légifrance</a></span> <small style="line-height:1em;">(consulté le <time class="nowrap" datetime="2020-02-08" data-sort-value="2020-02-08">8 février 2020</time>)</small></span>.</span>
</li>
<li id="cite_note-jep/07-01-3"><span class="reference-text"><abbr class="abbr indicateur-langue" title="Langue : anglais">(en)</abbr> Michael K. Bergman,
<a rel="nofollow" class="external text" href="http://www.press.umich.edu/jep/07-01/bergman.html">«&nbsp;<span class="lang-en" lang="en">The Deep Web: Surfacing Hidden Value</span>&nbsp;»</a>, <i><span class="lang-en" lang="en">The Journal of Electronic Publishing</span></i> 2001, <abbr class="abbr" title="volume">vol.</abbr>&nbsp;7, <abbr class="abbr" title="numéro">n<sup>o</sup></abbr>&nbsp;1.</span>
</li>
<li id="cite_note-4"><span class="mw-cite-backlink"><a href="#cite_ref-4">↑</a> </span><span class="reference-text"><span class="ouvrage" id="RennardZotto"><span class="ouvrage" id="Jean-Philippe_RennardPierre_Dal_Zotto"><abbr class="abbr indicateur-langue" title="Langue : anglais">(en)</abbr> Jean-Philippe <span class="nom_auteur">Rennard</span> et Pierre Dal <span class="nom_auteur">Zotto</span>, «&nbsp;<a rel="nofollow" class="external text" href="https://theconversation.com/darknet-darkweb-deepweb-ce-qui-se-cache-vraiment-dans-la-face-obscure-dinternet-128348"><cite style="font-style:normal;" lang="en">Darknet, darkweb, deepweb&nbsp;: ce qui se cache vraiment dans la face obscure d’Internet</cite></a>&nbsp;», sur <span class="italique">The Conversation</span> <small style="line-height:1em;">(consulté le <time class="nowrap" datetime="2020-02-10" data-sort-value="2020-02-10">10 février 2020</time>)</small></span></span>.</span>
</li>
<li id="cite_note-wright2009-5"><span class="mw-cite-backlink"><a href="#cite_ref-wright2009_5-0">↑</a> </span><span class="reference-text"><span class="ouvrage" id="Wright2009"><span class="ouvrage" id="Alex_Wright2009"><abbr class="abbr indicateur-langue" title="Langue : anglais">(en)</abbr> Alex <span class="nom_auteur">Wright</span>, «&nbsp;<cite style="font-style:normal" lang="en">Exploring a 'Deep Web' That Google Can’t Grasp</cite>&nbsp;», <i><span class="lang-en" lang="en">The New York Times</span></i>,‎ <time class="nowrap" datetime="2009-02-22" data-sort-value="2009-02-22">22 février 2009</time> <small style="line-height:1em;">(<a rel="nofollow" class="external text" href="https://www.nytimes.com/2009/02/23/technology/internet/23search.html?th&amp;emc=th">lire en ligne</a>, consulté le <time class="nowrap" datetime="2009-02-23" data-sort-value="2009-02-23">23 février 2009</time>)</small><span class="Z3988" title="ctx_ver=Z39.88-2004&amp;rft_val_fmt=info%3Aofi%2Ffmt%3Akev%3Amtx%3Ajournal&amp;rft.genre=article&amp;rft.atitle=Exploring+a+%27Deep+Web%27+That+Google+Can%E2%80%99t+Grasp&amp;rft.jtitle=The+New+York+Times&amp;rft.aulast=Wright&amp;rft.aufirst=Alex&amp;rft.date=2009-02-22&amp;rft_id=https%3A%2F%2Fwww.nytimes.com%2F2009%2F02%2F23%2Ftechnology%2Finternet%2F23search.html%3Fth%26emc%3Dth&amp;rfr_id=info%3Asid%2Ffr.wikipedia.org%3AWeb+profond"></span></span></span>.</span>
</li>
<li id="cite_note-6"><span class="mw-cite-backlink"><a href="#cite_ref-6">↑</a> </span><span class="reference-text"><span class="ouvrage">«&nbsp;<a rel="nofollow" class="external text" href="https://www.legifrance.gouv.fr/affichTexte.do?cidTexte=JORFTEXT000035638782&amp;categorieLien=id"><cite style="font-style:normal;">Vocabulaire de l'informatique et de l'internet (liste de termes, expressions et définitions adoptés)</cite></a>&nbsp;», sur <span class="italique">www.legifrance.gouv.fr</span> <small style="line-height:1em;">(consulté le <time class="nowrap" datetime="2020-02-09" data-sort-value="2020-02-09">9 février 2020</time>)</small></span>.</span>
</li>
<li id="cite_note-7"><span class="mw-cite-backlink"><a href="#cite_ref-7">↑</a> </span><span class="reference-text"><a rel="nofollow" class="external text" href="http://www.journaldunet.com/solutions/expert/65386/fraudes-en-ligne---ne-pas-ignorer-dark-web-et-deep-web.shtml">Fraudes en ligne&nbsp;: ne pas ignorer dark web et deep web </a>, sur <i>JournalDuNet</i>.</span>
</li>
<li id="cite_note-8"><span class="mw-cite-backlink"><a href="#cite_ref-8">↑</a> </span><span class="reference-text"><a rel="nofollow" class="external text" href="https://www.lemonde.fr/pixels/article/2015/10/01/plusieurs-sites-de-vente-de-drogue-du-deep-web-francais-pirates_4780425_4408996.html">Plusieurs sites de vente de drogue du «&nbsp;Deep Web&nbsp;» français piratés</a>, sur <i>LeMonde.fr</i>.</span>
</li>
<li id="cite_note-9"><span class="mw-cite-backlink"><a href="#cite_ref-9">↑</a> </span><span class="reference-text"><a rel="nofollow" class="external text" href="https://www.illicit-trade.com/fr/2018/06/red-rooms-dark-net-deep-web">Les «&nbsp;Red Rooms&nbsp;» du deep web: du mythe à la réalité</a>, 7 juin 2018, par Valentine Leroy</span>
</li>
<li id="cite_note-10"><span class="mw-cite-backlink"><a href="#cite_ref-10">↑</a> </span><span class="reference-text"><a rel="nofollow" class="external text" href="http://www.lepoint.fr/monde/deux-plaques-tournantes-du-dark-web-fermees-apres-une-operation-policiere-internationale-20-07-2017-2144659_24.php">Deux plaques tournantes du "Dark web" fermées après une opération policière</a>, sur <i>LePoint.fr</i>.</span>
</li>
<li id="cite_note-11"><span class="mw-cite-backlink"><a href="#cite_ref-11">↑</a> </span><span class="reference-text"><a rel="nofollow" class="external text" href="https://www.boursedirect.fr/fr/actualites/categorie/police-et-justice/deux-plaques-tournantes-du-dark-web-fermees-apres-une-operation-policiere-internationale-afp-c917a551867a6b6c3c44bf34e94431ccf56da7ae">Deux plaques tournantes du "Dark web" fermées après une opération policière</a>, sur <i>BourseDirecte.fr</i>.</span>
</li>
<li id="cite_note-12"><span class="mw-cite-backlink"><a href="#cite_ref-12">↑</a> </span><span class="reference-text"><a rel="nofollow" class="external text" href="http://www.rtl.be/info/magazine/hi-tech/on-a-presque-achete-des-armes-de-la-drogue-et-un-passeport-sur-internet-plongee-inedite-au-coeur-du-dark-web-902327.aspx">On a (presque) acheté des armes, de la drogue et un passeport sur internet&nbsp;: plongée inédite au cœur du DARK WEB</a>, sur <i>RTL.be</i>.</span>
</li>
<li id="cite_note-13"><span class="mw-cite-backlink"><a href="#cite_ref-13">↑</a> </span><span class="reference-text"><span class="ouvrage">«&nbsp;<a rel="nofollow" class="external text" href="http://www.ginjfo.com/actualites/divers/web-4-seulement-du-contenu-est-visible-ou-se-cache-le-deep-web-20150528"><cite style="font-style:normal;">Web, 4% seulement du contenu est visible, où se cache le Deep Web&nbsp;? - GinjFo</cite></a>&nbsp;», sur <span class="italique">GinjFo</span> <small style="line-height:1em;">(consulté le <time class="nowrap" datetime="2017-04-08" data-sort-value="2017-04-08">8 avril 2017</time>)</small></span>.</span>
</li>
<li id="cite_note-14"><span class="mw-cite-backlink"><a href="#cite_ref-14">↑</a> </span><span class="reference-text">Francis Pisani et Dominique Piotet, <i>Comment le web change le monde&nbsp;: l'alchimie des multitudes</i>, &nbsp;<abbr class="abbr" title="édition">éd.</abbr> Pearson, 2008 <small style="line-height:1em;">(<a href="International_Standard_Book_Number" title="International Standard Book Number">ISBN</a>&nbsp;<span class="nowrap">978-2-7440-6261-2</span>)</small>, <abbr class="abbr" title="page">p.</abbr>&nbsp;188.</span>
</li>
<li id="cite_note-15"><span class="mw-cite-backlink"><a href="#cite_ref-15">↑</a> </span><span class="reference-text"><abbr class="abbr indicateur-langue" title="Langue : anglais">(en)</abbr> Chris Sherman et Gary Price, <i><span class="lang-en" lang="en">The Invisible Web</span></i>, septembre 2001</span>
</li>
<li id="cite_note-16"><span class="mw-cite-backlink"><a href="#cite_ref-16">↑</a> </span><span class="reference-text"><span class="ouvrage"><abbr class="abbr indicateur-langue" title="Langue : anglais américain">(en-US)</abbr> «&nbsp;<a rel="nofollow" class="external text" href="https://googlewebmastercentral.blogspot.fr/2014/05/understanding-web-pages-better.html"><cite style="font-style:normal;" lang="en-us">Understanding web pages better</cite></a>&nbsp;», sur <span class="italique">Official Google Webmaster Central Blog</span> <small style="line-height:1em;">(consulté le <time class="nowrap" datetime="2016-03-08" data-sort-value="2016-03-08">8 mars 2016</time>)</small></span>.</span>
</li>
<li id="cite_note-17"><span class="mw-cite-backlink"><a href="#cite_ref-17">↑</a> </span><span class="reference-text"><span class="ouvrage"><abbr class="abbr indicateur-langue" title="Langue : anglais">(en)</abbr> «&nbsp;<a rel="nofollow" class="external text" href="http://www.seroundtable.com/archives/006665.html"><cite style="font-style:normal;" lang="en">Can A Search Engine Like Google.com Index My PDF Files?</cite></a>&nbsp;»</span>.</span>
</li>
<li id="cite_note-18"><span class="mw-cite-backlink"><a href="#cite_ref-18">↑</a> </span><span class="reference-text"><span class="ouvrage"><abbr class="abbr indicateur-langue" title="Langue : anglais">(en)</abbr> «&nbsp;<a rel="nofollow" class="external text" href="http://acrobatusers.com/tutorials/make-your-pdfs-work-well-google-and-other-search-engines"><cite style="font-style:normal;" lang="en">Make your PDFs work well with Google (and other search engines)</cite></a>&nbsp;»</span>.</span>
</li>
<li id="cite_note-19"><span class="mw-cite-backlink"><a href="#cite_ref-19">↑</a> </span><span class="reference-text"><span class="ouvrage"><abbr class="abbr indicateur-langue" title="Langue : anglais">(en)</abbr> «&nbsp;<a rel="nofollow" class="external text" href="https://support.google.com/webmasters/answer/72746?hl=en#1"><cite style="font-style:normal;" lang="en">Webmaster Tools Help&nbsp;: Flash and other rich media files</cite></a>&nbsp;»</span>.</span>
</li>
<li id="cite_note-20"><span class="mw-cite-backlink"><a href="#cite_ref-20">↑</a> </span><span class="reference-text"><span class="ouvrage" id="Pinte2011"><span class="ouvrage" id="Jean-Paul_Pinte2011">Jean-Paul Pinte, «&nbsp;<cite style="font-style:normal">Le Web invisible&nbsp;: l'antre du cybercrime</cite>&nbsp;», <i><a href="Pour_la_science" title="Pour la science">Pour la science</a></i>, <abbr class="abbr" title="numéro">n<sup>o</sup></abbr>&nbsp;70,‎ <time class="nowrap" datetime="2011" data-sort-value="2011">janvier-mars 2011</time>, <abbr class="abbr" title="page">p.</abbr>&nbsp;102<span class="Z3988" title="ctx_ver=Z39.88-2004&amp;rft_val_fmt=info%3Aofi%2Ffmt%3Akev%3Amtx%3Ajournal&amp;rft.genre=article&amp;rft.atitle=Le+Web+invisible+%3A+l%27antre+du+cybercrime&amp;rft.jtitle=Pour+la+science&amp;rft.issue=70&amp;rft.aulast=Pinte&amp;rft.aufirst=Jean-Paul&amp;rft.date=2011&amp;rft.pages=102&amp;rfr_id=info%3Asid%2Ffr.wikipedia.org%3AWeb+profond"></span></span></span>.</span>
</li>
<li id="cite_note-21"><span class="mw-cite-backlink"><a href="#cite_ref-21">↑</a> </span><span class="reference-text"><span class="ouvrage" id="Pinte2011"><span class="ouvrage" id="Jean-Paul_Pinte2011">Jean-Paul Pinte, «&nbsp;<cite style="font-style:normal">Le Web invisible&nbsp;: l'antre du cybercrime</cite>&nbsp;», <i><a href="Pour_la_science" title="Pour la science">Pour la science</a></i>, <abbr class="abbr" title="numéro">n<sup>o</sup></abbr>&nbsp;70,‎ <time class="nowrap" datetime="2011" data-sort-value="2011">janvier-mars 2011</time>, <abbr class="abbr" title="page">p.</abbr>&nbsp;103<span class="Z3988" title="ctx_ver=Z39.88-2004&amp;rft_val_fmt=info%3Aofi%2Ffmt%3Akev%3Amtx%3Ajournal&amp;rft.genre=article&amp;rft.atitle=Le+Web+invisible+%3A+l%27antre+du+cybercrime&amp;rft.jtitle=Pour+la+science&amp;rft.issue=70&amp;rft.aulast=Pinte&amp;rft.aufirst=Jean-Paul&amp;rft.date=2011&amp;rft.pages=103&amp;rfr_id=info%3Asid%2Ffr.wikipedia.org%3AWeb+profond"></span></span></span>.</span>
</li>
</ol></div>
</div>
<div class="mw-heading mw-heading2"><h2 id="Voir_aussi">Voir aussi</h2></div>
<div class="mw-heading mw-heading3"><h3 id="Articles_connexes">Articles connexes</h3></div>
<ul><li><span class="lang-en" lang="en"><a href="Gopher" title="Gopher">Gopher</a></span></li>
<li><span class="lang-en" lang="en"><a href="Darknet" title="Darknet">Darknet</a></span></li>
<li><span class="lang-en" lang="en"><a href="Dark_web" title="Dark web">Dark web</a></span></li></ul>
<div class="mw-heading mw-heading3"><h3 id="Liens_externes">Liens externes</h3></div>
<ul><li>Christophe Asselin, <a rel="nofollow" class="external text" href="http://c.asselin.free.fr/french/invisible_web.htm"><i>Web invisible, web caché, web profond</i></a></li>
<li><a rel="nofollow" class="external text" href="http://ptaff.ca/blogue/index.php/2006/03/31/comment_dacvoiler_le_web_cachac_gracce_a"><i>Mettre à jour le web invisible</i></a>, <i><a href="Le_Grand_Dictionnaire_terminologique" class="mw-redirect" title="Le Grand Dictionnaire terminologique">Le Grand Dictionnaire terminologique</a></i></li>
<li>Jean-Pierre Lardy, <a rel="nofollow" class="external text" href="http://www.addnb.fr/article.php3?id_article=35"><i>Le web invisible</i></a>, 2003, Université Claude Bernard - URFIST.</li>
<li><a rel="nofollow" class="external text" href="http://bibliotheque.unice.fr/services-et-formations/aide-et-formation/documents/Memo_WebInvisible.pdf"><i>Le web invisible</i> <abbr class="abbr indicateur-format format-pdf" title="Document au format Portable Document Format (PDF)">[PDF]</abbr></a>, 2011, Université Nice Sophia Antipolis.</li></ul>
<ul id="bandeau-portail" class="bandeau-portail"><li><span class="bandeau-portail-element"><span class="bandeau-portail-icone"><span class="noviewer" typeof="mw:File"></span></span> <span class="bandeau-portail-texte">Portail d’Internet</span> </span></li> </ul></div><!--htdig_noindex--><div><div class="zim-footer">
Cet article est issu de <a class="external text" title="Dernière modification le 2025-10-03" href="https://fr.wikipedia.org/wiki/?title=Web_profond&amp;oldid=229465411">Wikipédia</a>. Sauf mention contraire, le texte est disponible sous <a class="external text" href="https://creativecommons.org/licenses/by-sa/4.0/deed.fr">Creative Commons Attribution-Share Alike 4.0</a>. Des conditions supplémentaires peuvent s’appliquer aux fichiers multimédias.
</div>
</div><!--/htdig_noindex--></div>
</div>
</main>
</div>
</div>
</div>
<script src="./_webp_/webpHandler.js"></script>

</body></html>